메뉴

#학습 데이터

HN
Hacker News • 9일 전
IMP 5

쇼 HN: 당신의 AI는 얼마나 오래됐나? 20개 모델의 출시 시점과 학습 데이터 컷오프

개발자 Pawel Jozefiak이 주요 AI 모델 20개의 출시 후 경과 일수와 학습 데이터 컷오프(학습 중단 시점)를 자동 집계하는 정적 웹페이지를 공개했습니다. 모델은 출시일과 별개로 학습이 중단된 시점 이후의 정보를 알지 못하며, 웹 검색 도구는 이 간극을 임시로 덮어줄 뿐 근본적으로 해결하지 못한다는 점을 강조합니다. 모델에 컷오프 날짜를 직접 묻고, 날짜가 중요한 질문에는 검색을 켜라는 실용적 조언도 담고 있습니다.

모델 컷오프 AI 시계열 학습 데이터
TC
TechCrunch AI • 22일 전
IMP 7

메타, 신규 AI 모델 사용 데이터 제공 시 최대 95% 할인

메타가 새 AI 모델 '뮤즈 스파크(Muse Spark)'의 프롬프트와 출력 데이터를 공유하는 사용자에게 평균 약 95%의 요금 할인을 제공한다. 이는 사용자 데이터 확보에 어려움을 겪는 메타가 기업들에게 명시적인 보상을 제공해 학습 데이터를 확보하려는 전략으로, 프론티어 AI 기업 간 가격 경쟁과도 맞물려 주목된다.

메타 뮤즈 스파크 AI 가격 정책
TD
The Decoder • 57일 전
IMP 8

전 OpenAI 연구원 “단순 확장 한계…100조 원은 훈련 데이터로 간다”

전 OpenAI 연구원 앤드류 호는 단순히 대형 언어 모델(LLM)의 규모를 키우는 것만으로는 진정한 범용 성능을 낼 수 없다고 판단하여, 고품질 학습 데이터 제작 스타트업을 설립했습니다. 이는 경제적 가치가 높은 실무 작업들을 현재 AI가 제대로 수행하지 못하며, 향후 1,000억 달러(약 134조 원) 이상이 의미 있는 데이터 수집에 투자될 것이라는 전망에 기인합니다. 케임브리지대학교 및 구글 딥마인드 연구진 또한 최신 AI 모델들이 범용성보다는 특정 분야에 특화되고 있으며, 창의적 문제 해결에 한계에 직면했다는 분석으로 이를 뒷받침하고 있습니다.

대형 언어 모델 학습 데이터 일반화 한계
TC
TechCrunch AI • 100일 전
IMP 8

오픈AI도 주목하는 로봇 학습 데이터, XDOF의 700억 규모 도전

최근 AI 로봇 분야의 가장 큰 병목 현상은 언어 모델을 능가하는 고품질 '물리적 상호작용 데이터'의 부족입니다. 스타트업 XDOF는 원격 조종, 데이터 정제 및 파이프라인 구축을 전담하는 인프라 기업으로서 7천만 달러(약 950억 원)를 투자받았습니다. UC 버클리와 협력하여 역대 최대 규모의 로봇 훈련 데이터셋인 ABC를 공개하며, 선도적 AI 연구소들의 로봇 모델 학습을 가속화하고 있습니다.

로봇 공학 학습 데이터 XDOF
TD
The Decoder • 150일 전
IMP 9

엔비디아 네모트론 3 나노 옴니 공개

엔비디아가 텍스트, 이미지, 비디오, 오디오를 동시에 처리하는 오픈소스 멀티모달 모델 '네모트론 3 나노 옴니(Nemotron 3 Nano Omni)'를 공개했습니다. 이 모델은 경쟁사 모델(Qwen, GPT 등)에서 생성한 합성 데이터와 자체 오디오 데이터셋을 포함한 7,170억 개의 토큰으로 학습되었으며, 에이전트 애플리케이션에 최적화되어 상업적 사용이 가능합니다. 가장 주목할 점은 모델 가중치뿐만 아니라 학습 데이터, 파이프라인, 강화 학습 레시피까지 투명하게 공개하여 오픈소스 생태계에 큰 의미를 갖는다는 것입니다.

엔비디아 멀티모달 오픈소스